AIBase
首页
AI 资讯
AI 产品库
GEO 平台
MCP 服务
模型算力广场
VIP会员
ZH

AI资讯

查看更多

Meta 首个实时音频感知模型来了:20 多人同时说话也能分轨转写,每千分钟 3 美元

Meta推出首个实时音频感知模型Muse Voice Transcribe,可通过Model API调用,定价每1000分钟3美元(约每小时0.18美元)。该模型整合流式语音识别、说话人分离与端点检测,支持边说边转写,无需等待整段音频,并可自动区分20余名说话者分轨输出。

17.7k 31 分钟前
Meta 首个实时音频感知模型来了:20 多人同时说话也能分轨转写,每千分钟 3 美元

模型

查看更多

kimi-thinking-preview

Moonshot

kimi-thinking-preview

$200

输入tokens/百万

$200

输出tokens/百万

131

上下文长度

MCP

查看更多
NijiVoice

NijiVoice

NijiVoice-MCP是一个开发中的项目,实现了与にじボイス(Niji Voice)API的Model Context Protocol (MCP)集成,使LLM能够通过MCP接口轻松调用にじボイ斯的语音合成功能,包括语音生成、声优列表获取和余额查询等。

python
11.9k
2.5分
AIBase
智启未来,您的人工智能解决方案智库
English简体中文繁體中文にほんご
友情链接:
AI Newsletters AI ToolsMCP ServersAI NewsAI MarketingLLM LeaderboardAI Ranking
© 2026AIBase
商务合作网站地图